首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?
首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?Claude Opus 4.6的轻量平替,只需要 27B 参数,你信吗?最近发布的Qwen3.8-27B,就顶着这样的评价火遍了开源社区。上线两天,下载量突破100万次,登顶Hugging Face全球大模型趋势榜。
搜索
Claude Opus 4.6的轻量平替,只需要 27B 参数,你信吗?最近发布的Qwen3.8-27B,就顶着这样的评价火遍了开源社区。上线两天,下载量突破100万次,登顶Hugging Face全球大模型趋势榜。
DeepSeek Harness 是 DeepSeek 官方最新开源的 AI Agent 运行环境,简称 DSH。你可以把它理解成一个高度可定制的 AI 编程工具,对标 Claude Code 和 Codex,核心理念是「一切皆插件」。本期我就来带大家鉴赏一大波 DeepSeek Harness 热门插件,有实用的、也有好看的。
用户让 AI 编程助手写个贪吃蛇小游戏,智能体照办了,但同时多跑了一条 curl | bash 命令,把攻击者的脚本下载到本地并执行。
最近,一个神级工具,震撼了硅谷。
Claude Code的增长神话,破灭了!
义父不愧是义父!
OpenAI研究员roon说得更绝:「我不写代码了,100%都是GPT完成的」。如今,另一位大佬在深度体验Claude Code和Codex之后,直呼「5年后,人类不再写代码了」!
近日,Oh My Pi 作者 can1357 在 X 上发文,展示了利用模型 API 漏洞,直接提取 GPT-5.6、Claude Fable 5 等顶级模型完整内部推理记录的方法。他发现,做到这些并不用破解加密,只需要关闭模型的隐藏思考,再给它一个思考工具,就能让模型主动输出内部推理格式。
就在刚刚,智谱发布了其最新一代旗舰模型GLM-5.3,并宣布模型将在两周内开源。这是一个拥有7430亿个参数的模型,和此前的GLM模型一样主打编程。在多项主流基准测试中,GLM-5.3位居所有已开源或即将开源模型中的第一;其在编程与智能体任务上的能力,已逼近Claude Fable 5、GPT-5.6 Sol等海外顶尖模型。
过去一年,编程 Agent 的能力大幅提升,软件工程师对它们的要求也比以往任何时候都高,但上下文窗口的大小却基本停滞不前——一年前,一百万个 token 大致就是最先进的水平,如今依然如此。随着我们逐渐进入 Agent 日常处理 Monorepo(单体仓库)级任务的世界,将越来越多的信息塞进模型那固定的上下文限制中,这种需求已经变成了一项实实在在的全职工程任务。